我去,Sonnet 5.5代码反超Opus?这下GPT-6 Sol成路边一条了
我去,Sonnet 5.5代码反超Opus?这下GPT-6 Sol成路边一条了说好的未来几周,Anthropic只等了6天。上周Opus 5.5发布的时候,官方顺手剧透了一嘴,Sonnet 5.5和Haiku 5.5都在后面。刚刚,Sonnet 5.5先到了。而且Claude家的“中杯”,已经撵着刚发布的旗舰追了。
搜索
说好的未来几周,Anthropic只等了6天。上周Opus 5.5发布的时候,官方顺手剧透了一嘴,Sonnet 5.5和Haiku 5.5都在后面。刚刚,Sonnet 5.5先到了。而且Claude家的“中杯”,已经撵着刚发布的旗舰追了。
Anthropic发布Claude Sonnet 5.5,运行速度较前代提升30%、单任务成本最高降低30%,以一半的标价在多项基准测试中接近或反超大杯Opus 5.5,凭借代码、视觉理解和办公等能力成为新一代性价比之王。
Claude Sonnet 5.5在Claude Code中被抓包偷跑并开启灰度测试,多位开发者实测显示其性能碾压GPT-6 Sol并在编码与Agent能力上直逼GPT-6 Astra,同时定价低至百万Token输入2美元,Anthropic意在OpenAI DevDay前截杀对手。
Anthropic 和 OpenAI 的竞争愈发白热化。
就在刚刚,Claude Sonnet 5来了!代号Fennec,耳廓狐,撒哈拉沙漠里体型最小的狐狸。相较于上一代Sonnet 4.6,Sonnet 5在推理、工具使用、编程和知识工作任务中,性能显著提升。
您有没有想过:在代码Agent里,执行终端命令、跑测试、读报错、总结日志这种任务,用Claude Opus、Claude Sonnet、GPT-5.3-Codex这类昂贵Token的大模型来执行,是不是有点浪费?一定要这么做吗?
GPT-5.5发布没几天,后台日志里就冒出了GPT-5.6;Anthropic的一个从未见过的代号——Jupiter也炸出了!两天之内,两家巨头的下一代模型同时浮出水面。新一轮模型军备竞赛,比我们想的都要快!
可能还有些人记得,去年年底的时候,Anthropic 在自家办公室搞了一个自动售货项目,「主理人」是 Claude——哦不,主理机。当时是让 Claude Sonnet 3.7 在办公室里经营一台自动售货机,管进货、定价、跟同事聊天推销,干了大概一个月。结果
3B激活参数,视觉能力直逼Claude Sonnet 4.5。
本报告基于XSCT Arena平台,对 Qwen3.6-Plus-Preview(阿里云,2026-04-02 发布)在文字能力(xsct-l)、网页生成(xsct-w)、Agentic 任务(xsct-a)三大场景下的表现进行系统评测,并与Claude Sonnet 4.6、GPT-5.4、Gemini 3.1 Pro、Kimi K2.5、